本周 AI 项目推荐:UXBench、MemLens、RoadmapBench…下一代模型,需要下一代 Benchmark
本周 AI 项目推荐:UXBench、MemLens、RoadmapBench…下一代模型,需要下一代 Benchmark我们最近在重新思考一件事:到底什么样的 Benchmark,才值得今天继续做?
搜索
我们最近在重新思考一件事:到底什么样的 Benchmark,才值得今天继续做?
公告显示,“妙时”(含AI奇遇)将于7月14日0时正式停止运营。目前,平台已停止新用户注册、充值及会员购买等服务。停运后,“妙时”将全面关闭所有功能。用户账号中剩余的妙时币、曲奇币、电波及会员费用,可于8月14日前通过邮件申请退款。
AI 教育创业里,最容易做成的产品,就是上传资料,生成笔记、题目和闪卡。这类产品很多,包括我们之前介绍过的 StudyFetch、NotebookLM、Quizlet、Knowt、Anki 的 AI 插件,都在解决类似问题。
OpenAI 的 tevfik 写了篇关于 loop engineering 的文章,开头那句我读完顿了一下。他说,他和 coding agent 协作,到现在大多还是同一个流程:我解释一个任务,等结果,审一遍,再发下一条指令。代码是 agent 写的,但我在后台还干着另一份活——我记着发生了什么、决定下一步做什么、判断这事到底完成没。
斯坦福胡佛研究所追踪了 DeepSeek 七篇论文背后 356 名研究者的完整职业轨迹。美国培养出的最优秀 AI 人才正在大规模回流中国,而中国本土管道已经能独立产出前沿模型的核心贡献者。
据悉,AI 推理芯片公司上海淬思科技有限公司(Trace Intelligence,以下简称“淬思”)近日完成孵化轮融资,砺思资本(Monolith)与启盈同创基金联合领投。本轮资金将用于首款面向智能体(Agent)推理的专用芯片研发与流片,以及核心团队扩充。
近期,在 LangChain 举办的智能体大会 Interrupt 上,吴恩达与 LangChain 创始人 Harrison Chase 进行了一场关于 AI Agent 的对谈。整场交流的核心并不是简单讨论 Agent 有多强,而是围绕一个更现实的问题展开:当 AI Agent 让软件开发变快之后,真正的瓶颈会转移到哪里?
2026 年 6 月 19 日,John Jumper 在 X 上宣布,自己将离开工作近九年的 Google DeepMind,在短暂休整后加入 Anthropic。随后,DeepMind CEO Demis Hassabis 也公开回复,感谢 Jumper 对 AlphaFold 和 AI for Science 的贡献。
我们相信,常驻型 (always-on) AI 助理的下一次飞跃,不在于把某一个模型单点调得更聪明,而在于扩展智能体的上下文 (Scaling Agent Context)—— 不断拓宽助理能够持续 "感知 — 推理 — 执行" 的范围,作为生活连接器连接用户的信息孤岛,直到它能接管用户的整个数字世界。
对于 AI 生成图像中可能存在的不自然伪影,我们是否不仅能够将其定位和解释,还能进一步对其进行修复,使图像恢复为更加真实、自然的视觉外观?围绕这一问题,来自北京大学等机构的研究者提出了 GenShield:一个统一的自回归框架,将 AI 生成图像检测 与 图像伪影修复 结合到同一个闭环中,实现从 “诊断” 到 “修复” 的一体化建模。